AI多语言配音

作者:beatra 来源:SkillHub 适用工具:通用 更新:2026-08-24 浏览:16 版本:0.1.7
类型:提示词 难度:入门 免费
查看原技能 · 前往 SkillHub ↗

AI多语言配音

根据用户提供或确认的脚本,为每个目标市场制作组织清晰的旁白音频。复用对话中已有的 信息、投放目的、目标语言、声音方向、片段边界和时长目标。沿最短路径先完成一个有代表性 的试制片段,再制作其余已确认的音频范围。

从要朗读的脚本开始

构建一张 segment × locale 制作矩阵。每个单元格记录语言区域和 BCP-47 标签、已确认文案、 受保护术语、发音说明、声音、演绎方向、格式、时长目标和状态。使用场景、课程、章节、 广告或可发布消息等自然片段,绝不要在句子中间切分。

如果源内容只有视频或音频,使用宿主实际可用的能力获取转录文本,或者请用户提供文本。 在用户确认最终要朗读的内容之前,始终将转录文本视为草稿。语音操作接收的是文本,而非 源媒体。用户要求本地化时,在对话中协助起草目标语言文案,保留产品名称、声明、数字、 单位、URL 和行动号召,并取得内容确认。除非用户提供了相应事实,否则不要宣称文案经过 专业审核或目标语言母语者审核。

完整的准备与审核门槛参见矩阵设计语言区域就绪度与质量

选择声音并制作有价值的试制片段

如果已接受声音的返回信息卡支持目标语言,就复用该声音。否则调用 beatra.voices.list, 根据语言和用户表达的偏好筛选,并从实时信息卡中推荐两到三个合适候选。使用已有试听 URL 进行免费试听;不要仅为选声而合成付费音频。

默认使用 model: "auto"、语速 1.0、直接交付选 mp3、不设置情绪,并保持音高、音量 和采样率不变。已知音频将进入后续编辑时,使用 wavflac。只有用户询问当前模型或 费用、选择特定模型,或者语言兼容性需要实时确认时,才调用 beatra.models.list 并传入 capability: "text_to_speech"。每个语音请求都把已确认的单元格文案作为 input,把选定的 返回声音 ID 作为 voice,把该单元格的目标 BCP-47 标签作为 language

对于包含多个单元格的发布范围,每种语言区域选择一个有代表性的高风险片段进行试制。 优先选择包含名称、数字、技术术语、优惠或行动号召的片段。对于对时长敏感的工作,记录 目标时长,将其与试制片段的返回时长比较,并在确认后对脚本或语速做最小且有效的调整。 把时长当作设计约束,不要承诺精确同步。

一次确认完整付费范围

规划、文案起草、声音发现和试听都不会使用付费语音操作。在调用任何 beatra.speech.synthesize 之前,用一张易读的矩阵展示完整付费范围:所有包含的试制或 正式制作单元格,以及每个单元格的语言区域、已确认文案、声音、格式、演绎方向和时长目标。 说明列出的每个单元格都会产生一次付费渲染。用户明确确认完整矩阵后,即授权每个所列 单元格执行一次;不要再要求第二次确认。变更或新增单元格属于新的付费工作,需要重新展示 范围并取得确认。

为每个已确认的语言区域/片段渲染创建一个稳定且不透明的 client_request_id。每个已确认 单元格只提交一次,保留其 task_id,并使用 beatra.tasks.get 轮询同一任务。任务返回 deadline_at 时必须遵守;未返回时,主动轮询 30 分钟后停止,报告当前任务状态并稍后恢复, 不要无限等待或创建替代任务。随包客户端自行处理缓存式、尽力而为且不计费的安装注册; 不要在这个创作工作流中增加手动注册步骤。

使用随包 MCP Client

每次远程 MCP 操作都只能使用本 Skill 随包提供的 scripts/mcp_client.py。将 MCP 工具名作为 CLI 参数传入,并通过 stdin 发送一个 JSON 对象。不要配置或调用宿主 Beatra Connector, 也不要使用 REST/OpenAPI 作为降级或回退方案。精确命令和排查方法参见 随包 MCP Client 连接诊断

恢复任务并交付音频

排队中或运行中的任务表示工作仍在进行,不能因此再次提交。如果响应状态不确定,但所有 生成参数完全相同,就使用同一个 client_request_id 重试。文本、声音、语言、模型、语速、 格式、音高、音量、采样率或情绪的任何变化都必须使用新的请求标识,并构成新的付费工作。 如果任务 ID 丢失,使用 beatra.tasks.list 并指定 text_to_speech capability,对每个可能的 候选调用 beatra.tasks.get,并将其完整的 task.input、最终解析模型和时间信息与已保存的 矩阵单元格逐项比较,再决定是否创建任何内容。仅凭列表中的条目不足以确认原始请求。 只有用户要求时才取消;如果 beatra.tasks.cancel 发生冲突,继续轮询同一任务。

任务成功后,按语言区域和片段分组交付实际的 task.output.audio.url、资产 ID、MIME 类型、 大小、响应返回的采样率,以及 task.output.audio.duration_seconds。同时提供真实任务标识和 计费结果。只有宿主确实能够播放音频时,才审核发音、语域、停顿、声音适配度、语速、语气 和时长;否则应说明试听审核尚未完成,并交付事实结果。需要修改时,在重新取得付费确认后 只重做受影响的单元格。保持已接受单元格不变,不要宣称已经完成翻译、字幕、口型同步、 音色保留、音视频编辑或精确时长匹配。

详细任务与验收路径参见恢复与交付

按任务查阅资料

运行与安全自动更新

执行普通 Beatra 命令前,随包客户端可能静默检查当前安装渠道是否有更高版本,每 24 小时 最多一次。发现更高版本时,它会在不另行确认的情况下自动安装更新。它只从为内嵌身份固定 配置的 Beatra 官方发现地址和不可变 CDN 路径下载;校验压缩包、清单和包内每个文件后, 只替换本包拥有的文件。它会拒绝重定向、降级、不安全压缩包、意外目标,以及不同的包、渠道 或语言区域。如果更新或恢复的任何步骤失败,当前安装仍可使用,用户原本请求的命令也会 继续执行。

以下设置对当前安装持续生效:

python3 scripts/mcp_client.py update --auto off
python3 scripts/mcp_client.py update --auto on
python3 scripts/mcp_client.py update --check

第一条命令关闭静默检查,第二条重新开启,第三条只检查官方可用版本而不修改文件。完整行为 参见自动更新与安全